Skip to content
  • 0 Votes
    1 Posts
    32 Views
    A
    <p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-lungo.</p><p>Quando il contesto di una singola richiesta supera 272K token, l'input, la lettura della cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non rappresenta un aumento temporaneo o un addebito anomalo da parte di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale sarà comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e alle altre configurazioni di fatturazione.</p><p></p><p>La comparsa del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto lungo. Questo contrassegno indica principalmente che l'input e la lettura della cache sono passati a uno scaglione superiore; non significa che tutti i costi dell'intera richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore a scaglioni diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M indicata nell'articolo originale:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è effettivamente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma oltre 272K la fatturazione seguirà i prezzi dello scaglione superiore di OpenAI.</p><p></p><p>Per la configurazione originale, consultare: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-esteso.</p><p>Quando il contesto di una singola richiesta supera i 272K token, gli input, le letture dalla cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non da un aumento temporaneo dei prezzi o da un addebito anomalo di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale viene comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e alle altre impostazioni di fatturazione.</p><p></p><p>La presenza del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto esteso. Il contrassegno indica principalmente che l'input e la lettura dalla cache sono entrati in uno scaglione più elevato; non significa che tutti i costi dell'intera richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore a scaglioni diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M indicata nell'articolo originale:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è realmente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma i token oltre 272K verranno fatturati secondo i prezzi dello scaglione superiore di OpenAI.</p><p></p><p>Per la configurazione originale, consultare: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>
  • 0 Votes
    1 Posts
    78 Views
    A
    <p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-esteso.</p><p>Quando il contesto di una singola richiesta supera 272K token, l'input, la lettura della cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non rappresenta un sovrapprezzo temporaneo o un addebito anomalo da parte di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale viene comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e ad altre impostazioni di fatturazione.</p><p></p><p>La presenza del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto esteso. Il contrassegno indica principalmente che l'input o la lettura della cache sono entrati in uno scaglione superiore; non significa che tutti i costi della richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M dell'articolo precedente:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è effettivamente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma la parte oltre 272K verrà fatturata secondo gli scaglioni di prezzo più elevati di OpenAI.</p><p></p><p>Per la configurazione originale, fare riferimento a: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>